单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!
单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
搜索
本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
学不过来,刚刚学会怎么用好 Codex,现在又来了个 DeepSeek Harness。 过去几天,我们已经介绍过它的插件、各种新玩法和新上线的多模态,但还有一个最基础的问题没有解决:DeepSeek
DeepSeek 终于「开眼」了。就在刚刚,DeepSeek 推出了一款面向 Agent 时代的多模态模型:deepseek-v4-flash-vision-exp。目前,该模型已经上线 DeepSeek API 平台上,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。
DeepSeek Harness 是 DeepSeek 官方最新开源的 AI Agent 运行环境,简称 DSH。你可以把它理解成一个高度可定制的 AI 编程工具,对标 Claude Code 和 Codex,核心理念是「一切皆插件」。本期我就来带大家鉴赏一大波 DeepSeek Harness 热门插件,有实用的、也有好看的。
一个 Skill,就能让 DeepSeek V4 Pro 超过 Fable 5?
今天想和你聊聊 DeepSeek Harness。
前两天,DeepSeek 发布了 DeepSeek Harness。
太猛了,DeepSeek Harness 截至当前已经 112 k 的 Star 了,而这距发布仅仅过去三天。而且还在以惊人的速度增长...DeepSeek Harness 的核心就是:一切皆插件。说个不确切的比喻,有点 Agent 时代的 Obsidian 感觉了,自由度太高了。
DeepSeek-v4-pro-0813 正式上线,两极分化的口碑却让人摸不着头脑。一边,是疯狂刷屏的评测夯爆了:多项 Agent 测试逼近 Fable 5,被认为是又一次前沿模型的“核弹级”更新;另一边,却是不少深夜忠实开发者直摇头:吐槽涨价、模型能力不及预期,实测体感甚至不如之前的小模型……
今天凌晨,DeepSeek V4 Pro 正式版发布,引发热潮。现在,半天过去,DeepSeek Harness (开发者预览版)也来了!当然,这并不意外,毕竟该项目之前已经铺垫了很久了,比如 DeepSeek Harness 团队的崔添翼就一直在社交网络上发预热贴以及为该团队招募人才。